메뉴

#실시간 추론

HN
Hacker News 48일 전
IMP 9

디퓨전 젬마: 기존 대비 4배 빠른 텍스트 생성

구글이 텍스트를 병렬로 동시 생성하는 오픈소스 모델 'DiffusionGemma(디퓨전 젬마)'를 공개했습니다. 기존의 순차적 토큰 생성 방식을 탈피하여 단일 GPU에서 초당 1,000개 이상의 토큰을 생성하며, 고성능 소비자용 GPU에서도 원활하게 구동되는 것이 특징입니다. 양방향 어텐션(Bi-directional attention) 메커니즘을 통해 자가 교정 및 코드 삽입과 같은 비선형 텍스트 작업에 강점을 발휘하여 실시간 AI 애플리케이션 개발에 중요한 역할을 할 전망입니다.

디퓨전 모델 대형 언어 모델 (LLM) 오픈소스 AI
HN
Hacker News 54일 전
IMP 8

노트북으로 즐기는 오픈소스 실시간 AI 음악 모델

구글의 Magenta 팀이 실시간으로 반응하는 오픈소스 AI 음악 모델인 Magenta RealTime 2(MRT2)를 공개했습니다. 이전 버전과 달리 고성능 TPU/GPU 없이도 Apple Silicon 기반 맥북에서 매우 낮은 지연 시간(200ms)으로 작동하며, MIDI, 텍스트, 오디오를 통한 정밀한 제어가 가능합니다. 또한 C++ 기반의 고속 추론 엔진과 Python 라이브러리를 함께 제공하여 누구나 자신만의 AI 악기를 구축하고 DAW에 통합할 수 있습니다.

AI 음악 생성 실시간 추론 오픈소스 모델
TD
The Decoder 82일 전
IMP 8

오픈AI 실시간 음성 모델, GPT-5 수준 추론 능력 탑재

오픈AI가 실시간 추론, 번역, 전사 기능에 특화된 3종的新 음성 모델(GPT-Realtime-2, Translate, Whisper)을 공개했습니다. 특히 핵심 모델인 GPT-Realtime-2는 기존 텍스트 모델과 비견되는 GPT-5 수준의 추론 능력과 12만 8천 토큰의 긴 문맥 처리 능력을 제공합니다. 이를 통해 개발자들은 단순한 질의응답을 넘어 도구 사용과 복잡한 문맥을 이해하는 수준 높은 실시간 음성 AI 에이전트를 구축할 수 있게 되었습니다.

음성 AI GPT-5 실시간 추론